#AI 智能體
輝達宣佈Groq 3 LPX全面投產,Vera Rubin推理效率數倍提升,SpaceXAI加碼智能體與太空AI
輝達稱,基於SemiAnalysis的AgentX工作負載、採用DeepSeek V4 Pro模型,Vera Rubin每兆瓦吞吐量最高達到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。SpaceXAI將採用Vera CPU加速下一代智能體AI應用,並擴大基於Vera Rubin的平台建設,SpaceXAI計劃將優化版Vera Rubin NVL72延伸至太空,用於首代Starmind AI衛星。 輝達正在加速把AI基礎設施的競爭,從傳統的模型訓練和推理性能,推進到圍繞智能體AI(Agentic AI)的Token生成速度、能耗和成本展開的新階段。 美東時間24日周一,輝達宣佈面向互動式AI推理的Groq 3 LPX正式全面投產。作為Vera Rubin平台的重要組成部分,Groq 3 LPX主打超低延遲Token生成,輝達稱,在Artificial Analysis測試中,搭載Gemma 4 31B模型、100,000 Token上下文時,Groq 3 LPX實現每秒3400個輸出Token,為該模型創下最高紀錄;針對智能體編程等低延遲工作負載,其響應速度最高達到最近競爭平台的4倍。 同時,輝達公佈Vera Rubin NVL72在真實智能體工作負載下的新測試結果:基於SemiAnalysis的AgentX工作負載、採用DeepSeek V4 Pro模型,Vera Rubin每兆瓦(MW)吞吐量最高達到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。輝達強調,智能體任務不同於傳統聊天或摘要,任務上下文會隨著數百個步驟不斷累積,甚至達到數十萬Token。
Google:《2026年智見AI未來:智能體時代的AI創業新圖景》
在基礎大模型能力以月為單位急劇演進的今天,全球人工智慧產業正經歷一場前所未有的範式轉移。當通用的基礎設施能力不斷吞噬上一代產品的生存空間,初創公司的核心價值究竟應當錨定在何處?由Google Cloud(Google雲)聯合Google for Startups共同發佈的深度行業報告《智見AI 未來:智能體時代的 AI 創業新圖景》,通過對話15位活躍於全球AI創新前沿的創始人與頂級風險投資人,為這一時代命題提供了全面而深刻的解答。 報告指出,當前AI產業正在由單一模型能力的比拚,全面邁入以智能體(Agent)和系統化應用為核心的新階段。基礎模型逐漸商品化與基礎設施化,而深入物理世界、紮根特定業務流程、建構資料閉環與極致使用者體驗,正成為創業者無法被替代的護城河。對於以全球化為視野的新一代創業團隊而言,“生而全球”(Born Global)不再是一句口號,而是在第一天就必須確立的天然起點。 模型商品化趨勢與應用層護城河的遷移 過去一年中,大模型能力表現出強烈的“商品化”(Commoditization)特徵。隨著不同研發陣營在預訓練與後訓練技術上的突破,頂尖基礎模型的差距正在被快速拉平,模型API的呼叫成本亦呈現指數級下降。這種變化在為應用層帶來結構性紅利的同時,也給淺層套殼應用帶來了毀滅性的打擊。那些僅依靠簡單提示詞工程(Prompt Engineering)或單一生產環節構築的產品,極易在基座模型的下一次版本更新中被直接“吞噬”。